Type: entity
Confidence: 0.70
Created: 2026-04-20
Updated: 2026-04-20
Tags: personNLPRLHFalignmentAI工程

Long Ouyang

概述

OpenAI 研究员,InstructGPT 论文的第一作者,推动了大语言模型的人类偏好对齐研究。

关键内容

  1. InstructGPT 论文(2022):作为第一作者发表《Training language models to follow instructions with human feedback》,展示使用 RLHF(基于人类反馈的强化学习)对齐大语言模型
  2. RLHF 流程:通过监督微调、奖励模型训练、PPO(近端策略优化) 优化三步流程,使模型输出更符合人类偏好。
  3. ChatGPT 前身InstructGPTChatGPT 的直接技术前身,其对齐方法成为大语言模型部署的标准实践。

来源

相关